[随波逐流]OCR识别工具 使用说明书
截图即识 · 本地离线 OCR · 表格 / 条码 / 翻译 / 水印 / 双层 PDF / 批量转换 一体化的桌面效率工具
一、软件简介
随波逐流 OCR 识别工具是一款免费、免安装的 Windows 桌面效率工具,常驻系统托盘、随叫随到。屏幕上看到的文字,框一下就能变成可编辑文本——无论是网页文章、PDF 报告、表格单据,还是二维码、代码截图,统统一键识别。
- 离线引擎,数据不出电脑:内置 本地识别核心,不联网也能识别,中文与中英混排效果好,敏感内容更放心。
- 一站集成,不再东拼西凑:识别之外,翻译、整理、缩进、替换、水印、压缩、取色、图床全在这一个窗口里,装一个顶一堆小工具。
- 识别只是开始:结果集中在主文本框中,直接编辑、翻译、排版、导出 txt,识别到的内容马上就能用。
默认使用本地离线引擎;也可在「配置」中填入百度 API Key,一键切换在线识别(适配离线效果不佳的特殊场景)。
和主流OCR工具做个对比
| 功能 | 本程序 V5 | Umi‑OCR | PandaOCR | TextIn | Text‑Grab | NormCap | ShareX | 天若OCR |
|---|---|---|---|---|---|---|---|---|
| 截图与标注 | ||||||||
| 截图热键 / 全局截图 | ✓ | ✓ | ✓ | — | ✓ | ✓ | ✓ | ✓ |
| 截图标注 (形状/文字/马赛克) | ✓ | — | — | — | — | — | ✓ | ✓ |
| 序号标注 (圆底数字递增) | ✓ | — | — | — | — | — | ✓ | — |
| 截图贴图 (钉屏) | ✓ | ✓ | ◐ | — | ✓ | — | ✓ | — |
| 忽略区域 (免误识别) | ✓ | ✓ | — | — | — | — | ◐ | — |
| 滚动截图拼长图 | ✓ | ◐ | — | — | — | — | — | — |
| 识别核心 | ||||||||
| 离线 OCR 引擎 | ✓ | ✓ | ◐ | —(云端) | ✓ | ✓ | — | ◐ |
| 多语言识别 | ✓ | ✓ | ◐ | ✓ | — | ◐ | — | ◐ |
| 超长/超宽图分块识别 | ✓ | ◐ | — | ✓ | — | — | — | — |
| 竖排/多栏版式还原 | ✓ | — | — | ✓ | — | — | — | — |
| GPU 免配置加速 | ✓ | ◐ | — | — | ✓ | — | — | — |
| 表格识别 → Excel | ✓ | ✓ | — | ✓ | — | — | — | ◐ |
| 二维码 / 条码识别 | ✓ | ✓ | ✓ | ◐ | — | ◐ | ✓ | ✓ |
| 二维码 / 条码生成 | ✓ | — | — | — | — | — | ✓ | — |
| 文档与效率工具链 | ||||||||
| 双层可搜索 PDF | ✓ | ✓ | — | ◐(云端收费) | — | — | — | — |
| PDF 批量转 TXT/DOCX+自动整理 | ✓ | — | — | ◐(云端) | — | — | — | — |
| PDF 压缩 / 加水印 / 转 Word | ✓ | — | — | ✓ | — | — | ◐ | — |
| 批量图片识别导出 | ✓ | ✓ | ◐ | ✓ | — | — | ✓ | ◐ |
| 翻译 | ✓ | ✓ | ✓ | ◐ | — | — | — | ✓ |
三步上手
- 启动程序(默认最小化到托盘或直接显示主窗口)。
- 按 F8(默认文字识别快捷键),屏幕变暗后按住鼠标左键框选要识别的区域,松开即自动识别。
- 识别结果出现在主文本框中,可直接编辑、复制、导出;按 F7 仅截图不识别。
二、软件特色
内置 识别离线引擎,断网照样识别,中文 / 中英混排效果好,完全免费不限量。
滚动截图自动拼接;数千像素高的超长图自动分块识别、去重合并,一次出完整文本。
框选表格直接还原为Excel 表格,保留行列结构。
一次框选可同时识别画面中的多个二维码 / 条形码,支持 QR、Data Matrix、PDF 417、EAN、Code 系列等 21 种码制(详见下表)。
PDF 转 DOCX、PDF 四档质量压缩;图片批量压缩(保持原格式 / JPEG / PNG、可限宽)。
吸取屏幕任意位置颜色,返回颜色值,设计 / 前端取色利器。
中英互译一键完成:长文自动分段、多引擎自动兜底,译文单独成框不混排。
一键排版:合并 OCR 断行、去字间空格、列表项独立成段、去除重复行,还支持多步撤销。
文字水印 7 项参数全可调(颜色 / 透明度 / 角度 / 间距 / 字号 / 平铺或单个 / 玻璃样式)。
图片一键上传免费图床并返回外链,发帖、分享、写文档直接引用。
扫描版 PDF 外观不变,叠加一层可搜索、可复制的文字——转出来的文件在 Word、浏览器里都能直接选中文字。
整个文件夹的 PDF 一起转 DOCX(默认、宋体 12 磅)或 TXT,电子版直取文字层秒出、扫描件自动 OCR 兜底;几十张图片批量识别导出 TXT / MD / CSV。
矩形 / 椭圆 / 箭头 / 画笔 / 荧光笔 / 文字 / 马赛克,工具选中后粘滞可连续绘制;序号徽章点击自动递增;Ctrl+拖拽框忽略区域防误识;截图可贴图钉屏对照。
简体中文、繁体中文、英文、日文内置同一离线模型免下载;韩语等更多语种在配置中按需下载(约 10MB,一次下载永久离线可用)。
特色功能详解
- 文字识别——50+ 语言、横竖排自动识别。支持 50 余种语种文本解析,覆盖中英日韩、多语种欧洲语言、小语种及部分少数民族文字;自动判断文本排版方向,横向、竖排文字无需手动切换模式、无需提前矫正图片,轻微模糊、反光、倾斜的素材也能精准识别。追求更高精度可取消勾选「本地识别」切换百度在线接口(Key 自备);
竖排繁体书法识别 竖排日文识别 多语种识别 手写便签识别 有独显的机器自动走 GPU 加速,没有也流畅。多语言按需下载(配置-OCR 引擎) - 全能截图——长图拼接 + 标注贴图一站式。勾上「滚动截图」后页面滚到哪拼到哪,长图自动接起来,配合超长图自动分块识别,多长的图都能吃下;拼接处有重复,「段落去重」顺手清掉。矩形、椭圆、箭头、画笔、荧光笔、文字、马赛克一应俱全;「序号标注」点击即放圆底数字徽章、自动递增、可拖动缩放,写步骤图省事;「忽略区域」框住水印头像防误识;「贴图」
截图标注工具(矩形/椭圆/箭头/序号…) 滚动截图进行中 把截图钉在屏幕上对照抄参数。滚动截图自动拼接结果 - 条码识别与生成——全码制覆盖、批量解析。覆盖 Code 128、Code 39、EAN-13、EAN-8、UPC-A、UPC-E、ITF、Codabar 及 QR Code、PDF 417、Data Matrix、Aztec 等;支持一图多码一次识别全部输出;对拍照畸变、轻微倾斜、反光、噪点、局部遮挡自动做图像预处理增强;识别结果输出原始码数据,方便对接业务校验、数据录入与批量解析;
拍照反光条码识别 Data Matrix 识别 MaxiCode 识别 多码混合一次识别 右键菜单生成条码 支持批量图片解码并导出结果。支持的条码类型 - 表格识别——图片一秒生成可编辑 Excel。自动定位图片内表格,还原行列、合并单元格结构,拍照、扫描件、截图均可识别,
表格识别——图片一秒变可编辑 Excel 日文竖排翻译 导出后无需手动录入排版。韩文翻译 - 在线翻译——识别即翻译。可对接识别后的文字直接翻译,省去复制粘贴;支持批量文本翻译,
快速完成资料、文档语种转换。在线翻译 - 文本整理——识别即成稿。「自动整理」把一行一断的原始结果合并成完整段落;「段落去重」专治滚动长图衔接处的重复内容;「自动缩进」管首行格式。三个勾全开,
文本整理——断行合并成段落 多语种长文翻译 识别结果基本不用再动手改。右键文本整理 - 图片水印——文字水印防盗用。水印内容、透明度、大小与排布方式均可自定义,支持全屏平铺与角落单水印,
水印配置(文字/透明度/角度/平铺) 保护图片版权。桌面贴图(钉屏对照) - PDF 工具——常用处理一站集成。批量转换:整个文件夹的 PDF 一起转 DOCX 或 TXT(默认 DOCX、宋体 12 磅),自带文字层的电子版直接秒出,扫描件自动逐页 OCR 兜底;同一页签还有双层可搜索 PDF(外观不变、全文可搜可复制)与一键压缩,
PDF 批量转换(DOCX/TXT/双层/压缩) 转换选项(自动整理/段落去重/缩进) 批量转换进行中 适配存档、上传、发布、打印场景。双层可搜索 PDF 页签 - 图片处理——批量识别 + 批量压缩。批量图片识别:整个文件夹的图一次跑完,进度实时可见、中途能停,跑完按单文件导出 TXT / MD / CSV / DOCX,离线引擎本地跑、敏感单据不出电脑;批量图片压缩:自定义压缩质量,肉眼画质损失很小前提下大幅减小体积,
批量图片识别——一文件夹的图一次跑完 压缩后可打包下载。批量图片压缩 - 屏幕取色——一键取色。拾取屏幕任意位置颜色,获取十六进制、RGB 色值并支持复制色号,UI 设计、调色、
屏幕取色 网页开发快速取用。取色结果(HEX/RGB 色值) - 智能版面整理——文档级还原,不止于文字。识别结果自动还原文档版面:两栏 / 多栏按正确阅读顺序输出,跨栏大标题不拆碎;竖排文字(古籍、题字、对联)从右到左逐列还原,竖排标点多配置精读自动挽回;勾选「剔除页眉页脚」自动剔除书页顶 / 底部的页眉页码;勾选「标题层级」(配置 → 整理设置)自动加 Markdown 标题前缀,一键导出结构化 .md 文档;表格识别结果以 Markdown 表格并入文本框、另存 Excel 双格式输出。
支持的条码类型(共 21 种)
| 1D 商品码 | 1D 工业码 | 2D 码 |
|---|---|---|
| UPC-A | Code 39 | QR Code |
| UPC-E | Code 93 | Data Matrix |
| EAN-8 | Code 128 | Aztec |
| EAN-13 | Codabar | PDF 417 |
| UPC/EAN Extension 2/5 | ITF | MaxiCode |
| Barcode | RSS-14 | |
| RSS-Expanded |
三、软件界面
| 区域 | 说明 |
|---|---|
| 顶部按钮栏 | 25 个功能按钮(鼠标悬停有浮框提示、高亮反馈):识别类 → 文本处理 → 文件 → 工具 → 系统。最左侧是软件图标,按住可拖动窗口。 |
| 主文本框 | 识别结果与编辑区,支持多步撤销(最多 20 步)。点击「显示/隐藏文本框」可收起整窗。 |
| 译文框 | 点击「在线翻译」后在右侧出现,含「复制 / 导出 / ✕ 关闭」。 |
| 底部勾选栏 | 9 个功能开关(详见第八节),展开文本框时显示。 |
| 更新提示行 | 有新版本时在文本框下方显示红色提示与「升级」按钮。 |
| 系统托盘 | 点 ✕ 关闭仅隐藏到托盘,双击托盘图标或按 Ctrl+F1 恢复。 |
四、按钮逐个介绍(从左到右)
按主界面上从左到右的实际排列顺序逐个介绍(序号即从左数第几个):
| 从左数 | 按钮 | 功能说明 |
|---|---|---|
| 第 1 个 | 文字识别 | 核心功能:框选屏幕区域识别为文字(快捷键 F8),默认本地离线引擎。 |
| 第 2 个 | 屏幕截图 | 仅截图不识别(快捷键 F7),截图进剪贴板。 |
| 第 3 个 | 条码扫码 | 框选二维码 / 条形码,解码结果直接写入文本框。 |
| 第 4 个 | 表格识别 | 框选表格区域输出 Excel 表格。 |
| 第 5 个 | 在线翻译 | 中英互译,译文显示在右侧译文框;长文自动分段、多引擎自动兜底(见第六节图 4)。 |
| 第 6 个 | 首行缩进 | 按「配置 → 缩进量」为段落首行加缩进(默认 2 全角空格)。 |
| 第 7 个 | 文本整理 | 一键排版:合并 OCR 断行、去字间空格、列表项独立成段、去除重复行。 |
| 第 8 个 | 文本替换 | 弹出查找 / 替换对话框,对文本框内容批量替换。 |
| 第 9 个 | 撤销 | 多步撤销(最多 20 步):替换、整理、清空、缩进等操作都能回退。 |
| 第 10 个 | 清空 | 清空文本框内容;误清可点「撤销」找回。 |
| 第 11 个 | 复制 | 一键复制文本框全部内容到剪贴板。 |
| 第 12 个 | 粘贴 | 先清空文本框,再贴入剪贴板内容——文字、截图均可(与右键粘贴的光标插入不同)。 |
| 第 13 个 | 上传图床 | 上传图片到免费图床并返回外链,方便发帖分享。 |
| 第 14 个 | 导入 | 把 .txt(自动识别编码)、.docx 或图片文件导入文本框;旧版 .doc 请先转存 .docx。 |
| 第 15 个 | 导出 | 把文本框全部内容保存为 txt / Markdown(.md)文件,图片保存为图片文件。 |
| 第 16 个 | 水印 | 按「配置」中的参数给图片加水印(文字 / 颜色 / 透明度 / 角度 / 间距 / 字号 / 平铺或单个 / 玻璃样式)。 |
| 第 17 个 | PDF 工具 | 四个页签:PDF 转 DOCX(转 Word 可编辑文档)、PDF 压缩(四档质量)、双层 PDF(外观不变叠加可搜索可复制文字层)、批量转换(整个文件夹转 DOCX / TXT / 双层 PDF,自动整理,扫描件自动 OCR 兜底)。基于内置 Ghostscript,无需另装组件。 |
| 第 18 个 | 图片压缩 | 批量压缩图片:保持原格式 / JPEG / PNG、压缩比滑块、可限定最大宽度。 |
| 第 19 个 | 批量图片识别 | 选一个文件夹,几十张图片一次跑完:进度实时可见、中途可停止;勾选「收缩时隐藏」后最小化不打扰工作。结果按单文件导出 TXT / Markdown / CSV(Excel 可开)。 |
| 第 20 个 | 屏幕取色 | 吸取屏幕任意位置颜色,返回颜色值,做设计 / 写网页常用。 |
| 第 21 个 | 配置 | 打开配置窗口:常规(启动最小化、快捷键、缩进量)、整理设置(段落去重、标题层级)、百度联网识别、水印全套参数、OCR 引擎(识别语言、GPU、阈值等),分五组排列。 |
| 第 22 个 | 赞赏 | 打开「赞赏作者」窗口,扫码支持作者。 |
| 第 23 个 | 帮助 | 打开在线帮助教程页(http://www.1o1o.xyz/bo_ocr.html)。 |
| 第 24 个 | 更新 | 手动检查新版本;发现新版本时文本框下方出现红色提示行与「升级」按钮。 |
| 第 25 个 | 显示/隐藏文本框 | 收起 / 展开文本区与底部勾选栏,让窗口缩成一行按钮,不遮挡工作区。 |
| 第 26 个 | ✕ 关闭 | 隐藏主窗口到系统托盘(并非退出),按 Ctrl+F1 或双击托盘图标恢复。 |
五、识别功能
| 功能 | 用法与说明 |
|---|---|
| 文字识别 F8 | 框选区域 → 识别为文本。勾选「本地识别」走离线引擎;取消勾选则调用百度在线接口(需在配置中填 API Key)。含智能排版:自动合并断行、去重复行、按语种补空格,并自动过滤低置信度的碎字噪声(保留长文本,不误删正文)。 |
| 多栏 / 竖排还原 | 两栏、多栏文档按「左栏读完读右栏」的正确阅读顺序还原,跨栏大标题自动先于正文输出;竖排文字(古籍、对联、题字)按从右到左逐列还原,竖排标点通过多配置精读自动挽回,不会整篇丢句读。 |
| 屏幕截图 F7 | 仅截图不识别,图片保存到剪贴板。截图后可用工具栏「贴图钉屏」把选区钉在桌面上。 |
| 截图标注 | 框选后可在选区内标注:矩形 / 椭圆 / 箭头 / 画笔 / 荧光笔 / 文字 / 马赛克。工具粘滞——选中后可连续绘制,直到切换工具或再次点击取消;序号标注点击放置圆形数字徽章、自动递增,可拖动移动、悬停滚轮缩放,撤销后序号自动回退。Ctrl+拖拽可框选忽略区域(红框标出,识别时剔除水印头像等)。标注会一并进入 OCR、保存与复制结果。 |
| 贴图钉屏 | 截图工具栏「贴图」按钮:把选区钉成置顶无边框小窗——按住拖动移动、滚轮缩放(光标位置不动)、双击或右键关闭,可同时钉多张。照着参考图抄参数、对照录入时很好用。 |
| 多语言识别 | 「配置 → OCR 引擎 → 识别语言」选择语种:简体中文+英文、繁体中文、日文内置同一离线模型免下载;韩语等更多语种首次选用需联网下载模型(约 10MB,一次下载永久离线可用)。 |
| 条码扫码 | 框选二维码 / 条形码,识别结果直接写入文本框。 |
| 表格识别 | 框选表格区域:结果以 Markdown 表格插入文本框(可直接复制进 Word / 笔记软件),同时弹出保存对话框另存 Excel(.xlsx)文件,双格式一次拿到。 |
| 滚动截图(勾选) | 开启后支持滚动拼接:多次截图自动上下拼接成超长图再识别。软件对超高长图(数千像素高)会自动分块识别并合并结果,无需手工切图。 |
六、文本处理
| 功能 | 用法与说明 |
|---|---|
| 在线翻译 | 把文本框内容中英互译,译文显示在右侧译文框。内置多个翻译接口。 |
| 文本整理 | 一键排版:合并 OCR 断行、清除 CJK 字间空格、列表项独立成段、去除重复行(数字归一化对比);保留段落间距(空行),一级 / 二级列表自动分级缩进。 |
| 标题层级(配置勾选) | 在「配置 → 整理设置」勾选「标题层级」后,识别时按行高聚类自动给标题行加 Markdown # / ## 前缀,配合「导出 → Markdown」可直接得到带层级的 .md 文档(导入 Typora、Obsidian 等笔记软件即为标准标题)。 |
| 首行缩进 | 按「配置 → 缩进量」所选单位(默认 2 全角空格)为段落首行加缩进。 |
| 文本替换 | 弹出「查找 / 替换」对话框,对文本框内容批量替换。 |
| 撤销 | 多步撤销(上限 20 步):替换、整理、清空等操作均可回退。 |
| 复制 / 粘贴 | 按钮「粘贴」= 先清空文本框再贴入剪贴板内容(文字或图片均可);右键「粘贴」= 在光标处插入,不动已有内容(详见第八节)。 |
| 清空 | 清空文本框(可撤销)。 |
七、文件与图片工具
| 功能 | 用法与说明 |
|---|---|
| 导入 | 把 .txt(自动识别编码)、.docx、常见图片导入文本框;旧版 .doc 请先转存 .docx。 |
| 导出 | 把文本框内容保存为 txt 或 Markdown(.md)文件——勾选「标题层级」后导出的 .md 自带 # 标题结构,可直接导入笔记软件。 |
| 上传图床 | 把图片上传到免费图床并返回外链;右键菜单也可对选区图片使用。 |
| 水印 | 对图片加水印:文字、颜色、透明度、角度、间距、字号、平铺 / 单个模式、玻璃磨砂样式均可在「配置」中调整(默认文字「随波逐流版权所有」、红色、50% 透明、-40°)。 |
| 图片压缩 | 批量压缩:选输入路径与输出目录,支持保持原格式 / JPEG / PNG,压缩比滑块、限定最大宽度。 |
| PDF 工具 | 四个页签:PDF 转 DOCX;PDF 压缩(四档质量);双层 PDF——逐页识别并叠加不可见文字层,外观不变、可搜索可复制;批量转换——整个文件夹转 DOCX(默认、宋体 12 磅)/ TXT / 双层 PDF,勾选「自动整理」连段落都排好,自带文字层的电子版秒出、扫描件自动逐页 OCR 兜底。基于内置 Ghostscript,无需另装组件。 |
| 批量图片识别 | 选文件夹批量识别:进度实时、中途可停、识别中可最小化;结果合并导出 TXT / Markdown / CSV(Excel 可开)。离线引擎本地运行,整批单据不出电脑。 |
| 屏幕取色 | 框选或点击屏幕任意位置取色,返回颜色值。 |
| 配置 / 更新 / 帮助 / 赞赏 | 配置见第九节;更新检查新版本;帮助打开在线教程页。 |
八、功能开关(底部勾选栏)
| 开关 | 作用 |
|---|---|
| 窗口置顶 | 主窗口始终保持在最前,不被其他窗口遮挡。 |
| 本地识别 | 勾选 = 本地离线 OCR;取消 = 百度在线识别(需配置 Key)。 |
| 追加识别 | 新识别内容追加到文本框末尾,不清空已有内容。 |
| 自动整理 | 识别完成后自动执行「文本整理」。 |
| 自动缩进 | 识别完成后自动执行「首行缩进」。 |
| 剔除页眉页脚 | 识别书页 / 文档扫描件时,按版面位置自动剔除页顶 / 页底带内的页眉、页脚、页码(如「第 12 页」「- 3 -」),正文不受影响;滚动长图不适用。配合「自动整理」使用,转档文档更干净。 |
| 滚动截图 | 启用滚动拼接长图模式。 |
| 自动水印 | 识别完成后自动按配置给图片加水印。 |
| 开机自启 | 通过启动项快捷方式实现开机自动运行;取消勾选即移除。 |
九、右键菜单
在主文本框上点右键:
| 菜单项 | 说明 |
|---|---|
| 复制 / 剪切 / 粘贴 | 常规剪贴板操作。注意:右键「粘贴」是光标处插入,与顶部按钮「粘贴」(先清空再贴)不同。 |
| 导入文件到文本框 / 导出文本框内容 | 同顶部「导入 / 导出」按钮。 |
| 截图文字识别 / 截图表格识别 | 临时框选识别,不打断当前内容。 |
| 百度文字搜索 / 必应文字搜索 | 把选中文本直接送去搜索引擎。 |
| 图片上传图床 | 上传文本框中的图片并复制外链。 |
| 二维码 / 条码生成 | 二级菜单选码制(QR Code、Data Matrix、Code 128、EAN-13 等),对选中文本(未选中则取全文)生成二维码 / 条码图片,可直接粘贴到聊天或文档。 |
十、配置窗口
配置窗口按功能分为五组:
1、常规(启动 / 快捷键 / 缩进)
| 配置项 | 说明 |
|---|---|
| 启动时最小化 | 勾选后启动驻留系统托盘、不弹主窗口,适合开机自启常驻场景。 |
| OCR 快捷键 / 截图快捷键 | 默认 F8 / F7,可改成 ctrl+f1、ctrl+alt+o 等组合。 |
| 缩进量 | 首行缩进的单位(默认 2 空格全角)。 |
2、整理设置(段落去重 / 标题层级)
| 配置项 | 说明 |
|---|---|
| 段落去重 | 勾选后,识别完成与手动「文本整理」时自动执行整块重复段落去重——专治滚动长图衔接区重复内容。注意:歌词等合法重复也会被删,请酌情勾选。 |
| 标题层级 | 勾选后,识别时按行高聚类给标题行自动加 Markdown # / ## 前缀,配合「导出 → Markdown」得到带层级的 .md 文档。 |
3、百度联网识别(仅未勾选「本地识别」时生效)
| API Key / Secret Key | 使用百度在线识别时必填。 |
4、水印
| 配置项 | 说明 |
|---|---|
| 水印文字 / 颜色 / 透明度 / 角度 / 间距 / 字号 | 水印内容与样式,颜色点选色器选取(默认颜色为灰色 #808080)。 |
| 平铺模式 | tile = 平铺整图;single = 图片中央单个水印。 |
| 玻璃样式 | 水印文字带磨砂半透明描边,更美观且不遮挡正文。 |
5、OCR 引擎(本地识别)
| 配置项 | 说明 |
|---|---|
| 识别语言 | 简体中文+英文、繁体中文、日文内置同一离线模型免下载;韩语等更多语种按需下载(约 10MB,一次下载永久离线可用)。 |
| 置信度阈值 | 低于阈值的结果被丢弃。改小可多认出模糊文字但易出错(默认 0.5)。 |
| 方向纠正 | 识别横排 / 180° 倒转文本(默认开)。 |
| 边长上限(px) | 送入识别引擎前图片最长边的缩放上限(默认 2000)。 |
| 计算模式 | 自动探测(推荐,有独显自动走 GPU)/ 强制 CUDA / 强制 DirectML / 仅 CPU。 |
十一、快捷键一览
| 快捷键 | 功能 |
|---|---|
| F8 | 文字识别(框选即识,可在配置中修改) |
| F7 | 屏幕截图(仅截图,可在配置中修改) |
| Esc | 取消当前框选 / 截图 |
| Ctrl+F1 | 从托盘恢复主窗口 |
| Ctrl+左键拖拽 | 截图时框选忽略区域(识别时剔除),可添加多个 |
| Ctrl+Z | 截图标注时撤销上一步标注 / 徽章 |
十二、常见问题
Q1:识别结果乱码 / 排版乱?
先点「文本整理」尝试自动修复;长图请确认已勾选「滚动截图」或使用滚动拼接,超高长图软件会自动分块处理。截取区域尽量贴合文字、避免过小的字号。
Q2:翻译失败或译文就是原文?
软件已内置多引擎级联与坏结果自动重试。若仍失败多为网络问题(部分引擎需要能访问外网),稍后重试即可;提示信息会写入日志。
Q3:程序关不掉了?
点 ✕ 是「隐藏到托盘」而非退出;双击托盘图标或按 Ctrl+F1 恢复后再从托盘图标右键退出。
Q4:出了问题怎么反馈?
程序目录下的 logging.log 记录了本次运行的全部信息(每次启动自动清空重建),反馈问题时请附上该文件。
Q5:在线识别报错?
检查配置中的百度 API Key / Secret Key 是否正确、账户是否有余额;不使用在线识别时保持「本地识别」勾选即可,完全免费离线。
Q6:日语 / 韩语识别不了?
到「配置 → OCR 引擎 → 识别语言」切换语种。简体中文、繁体中文、日文已内置同一离线模型,选中即用;韩语等更多语种首次选用会提示联网下载模型(约 10MB),下载一次永久离线可用。识别不出内容时会有空结果提示,请检查语言选择是否与图片一致。
Q7:扫描版 PDF 转出来能复制文字吗?
能。用「PDF 工具 → 双层 PDF」生成的文件外观不变,底层带可搜索、可复制的文字层;整个文件夹的 PDF 用「批量转换」页签一次转完(DOCX / TXT / 双层 PDF 可选,默认 DOCX)。
十三、关于本软件
- 软件名称:[随波逐流]OCR识别工具
- 在线帮助 / 最新版本:
http://www.1o1o.xyz/bo_ocr.html - 本软件为免费软件,如果觉得好用,欢迎点「赞赏」支持作者。
- 免费声明:本软件为永久免费软件,所有功能均可免费使用,不收取任何费用。如遇第三方以本软件名义进行收费售卖,均与本项目无关,请提高警惕、谨防受骗,下载请认准官方下载地址。
- 官方唯一地址:随波逐流安全信息网
1o1o.xyz;下载地址:http://www.1o1o.xyz/bo_ocr.html - 持续更新:本工具依托 AI 辅助开发,大型项目持续迭代会产生较高 Token 开销,个人维护压力较大。若工具对您有所帮助,欢迎自愿赞助支持持续更新——赞助完全自愿,不付费不影响软件全部功能使用。
- 这款工具从个人自用版本迭代至今,所有优化升级均来自真实用户反馈。始终坚持干净、免费、高效、无套路的初衷——不打扰、不收割、不泄露。